返回AI 可解释性

AI 可解释性

Anthropic
2026-07-17 07:37:09

J-Space 引发可解释性讨论:本体工程被提出为 AI 黑箱另一把钥匙

MarsBit刊发署名“ASI启示录”、来自微信公众号“新智元”的文章,围绕 Anthropic 研究团队 2026 年 7 月发表的《A global workspace in language models》展开讨论。文中介绍了通过 J 透镜识别 Claude 内部 J-Space 的研究进展,同时指出,把可解释性仅放在模型内部状态上存在内在主义、功能类比和工程化窄化等局限,并主张把解释重心转向信息本体论与本体工程,将模型输出锚定在可追溯的知识结构之上。

350
J-Space 引发可解释性讨论:本体工程被提出为 AI 黑箱另一把钥匙
Anthropic
2026-07-13 14:02:46

Anthropic J-Space 论文引发误读:可解释性工具不等于 AI 具有意识

Anthropic 7 月 6 日发布的 244 页 J-Space 论文,再次把“AI 是否有意识”的讨论推到台前。论文借助 J-lens 在 Claude 内部定位出一个占模型活动不到 10% 的推理子空间,并展示了它在安全监控和行为分析上的潜力。但论文同时明确表示,这一发现无法证明 AI 具备意识。文章认为,J-Space 更准确的定位是一种有价值但仍有局限的可解释性工具,而非“Claude 产生意识”的证据。

220
Anthropic J-Space 论文引发误读:可解释性工具不等于 AI 具有意识